跳到正文
#
拾穗
beta
登录
加入会员
最新
资讯
方法
观点
专题
职场认知
职业成长
商业洞察
数据工程
AI
数据分析
数据治理
求职面试
视听
播客
视频
知识库
专属
咨询
关于
#
拾穗
beta
最新
资讯
方法
观点
专题
视听
知识库
专属
咨询
关于
登录
加入会员
最新
资讯
方法
观点
专题
职场认知
职业成长
商业洞察
数据工程
AI
数据分析
数据治理
求职面试
视听
播客
视频
知识库
专属
咨询
关于
全部标签
apache iceberg
#
apache iceberg
共 3 篇文章
数据工程
·
方法
把数据湖换成 Iceberg 前,先找出最值得迁的 3 张表
Grab 把 Hive Parquet 迁往 Apache Iceberg 后,部分查询从约 70 秒降到 6 秒,部分 S3 API 成本最多下降约 95%。但普通数据开发不该先问要不要全湖迁移,而应从小文件、查询频率、元数据等待和人工补分区里找出最值得先动的 3 张表。
PRO
数据工程
·
方法
Iceberg 迁移决策表:从小文件、查询成本到回滚计划
团队准备从 Hive Parquet 迁往 Apache Iceberg 时,最容易缺的不是技术介绍,而是一张能比较收益、兼容性和回滚风险的决策表。本文给数据开发一套 Pro 模板,用 6 组指标筛选候选表,并把基线、试点、双读验证和退出条件写进迁移计划。
数据工程
·
资讯
数据周刊|Agent 开始改写数据库、图表和分析助手
Data Engineering Weekly #278 把 5 个信号放到了一起:Agent 可能一次发出上千条 SQL,Microsoft Flint 尝试让 AI 稳定生成图表,Grab 用 Apache Iceberg 处理海量小文件,AWS 重做 MCP 工具接口。普通数据开发和分析师该先补哪一层?
未在播放
✕
0:00
0:00
✕
喜欢这里的内容?
加入社区免费交流,或升级会员解锁全部深度内容。
免费加入社区
了解会员